谷歌突然发布“最强听写模型”:Agent时代的落伍产品,还是关键拼图?
谷歌突然发布“最强听写模型”:Agent时代的落伍产品,还是关键拼图?谷歌发布语音转文本模型Gemini 3.5 Transcribe,支持85种以上语言、流式转录与智能整理功能,流式词错误率为4.0%,文章认为该模型并非Agent时代的落伍产品,而是语音Agent走向生产环境所必需的关键基础拼图。
搜索
谷歌发布语音转文本模型Gemini 3.5 Transcribe,支持85种以上语言、流式转录与智能整理功能,流式词错误率为4.0%,文章认为该模型并非Agent时代的落伍产品,而是语音Agent走向生产环境所必需的关键基础拼图。
近日,Meta 首席 AI 官、被称为公司“最高薪员工”的 Alexandr Wang,因一句简单却极具挑衅意味的话引起热议:“gemini who?(Gemini,谁啊?)”这场口水战的背后,其实是一场 AI 巨头之间的公开较量——Meta 最新模型 Muse Spark 1.1 在一份模型排行榜中超过了谷歌刚发布的 Gemini 3.6 Flash
彭博社的一则独家报道如同一盆冰水,浇灭了所有人的热情:Gemini 3.5 Pro发布延期了,而且不是延期几天,是数月的大延期!本该是载入史册的发布,被谷歌自己按下了暂停。
最新消息终于来了——Gemini 3.5 Pro或将于7月17日正式上线。更有意思的是,这个日期恰好与国产大模型DeepSeek V4正式版的发布窗口正面重合。那么这一次,谷歌拿出的究竟是“真金”还是“虚火”?不妨从三个维度拆解一下。
今天,全网都被Gemini 3.5 Pro的泄露刷屏了。传闻中,7月17日正式发布。而真正让坐不住的,是它在前端生成上的表现:一次成型、像素级精准、零失误。最关键的是,Gemini 3.5 Pro性能爆出超越了Fable 5。
好好好,起大早赶晚集的谷歌,这次又拿出了新东西—— Computer use,就是那个电脑操作能力,这回直接被内置进Gemini 3.5 Flash:
谷歌留不住人了!诺奖得主离职后,Gemini两大核心将一同入职Anthropic。同一天,Gemini 3.5 Pro已延期至7月。
据最新独家爆料,谷歌目前正在紧锣密鼓地对即将发布的重磅大语言模型Gemini 3.5 Pro进行高强度的激进迭代,在正式揭晓之前,内部预计还会测试更多的版本。
刚刚,Google 甩出了 Gemini 3.5 Live Translate。这是它最新的语音对语音翻译模型,一句话概括:把「等你说完再翻」的老规矩,直接掀了。Google DeepMind 首席科学家 Jeff Dean 亲自发帖官宣,字里行间透着一股「二十年磨一剑」的底气:
普通人看排行榜估计越看越疑惑,写文章该用哪个?数据分析该用哪个?写代码、审 PR、拆任务又该用哪个?我挑了四款最近讨论度很高的模型:Claude Opus 4.8、Gemini 3.5 Flash、GPT-5.5、Qwen3.7-Max,做一次横评,看看它们在真实任务里的交付表现。